((Traduction automatisée par Reuters à l'aide de l'apprentissage automatique et de l'IA générative, veuillez vous référer à l'avertissement suivant: https://bit.ly/rtrsauto))
* SemiAnalysis a passé au crible 857 versions publiées par neuf grands développeurs chinois
* Seules neuf versions disposaient de rapports de sécurité publiés au moment de leur lancement
* Le rapport évalue la divulgation publique des résultats des tests, et non le fait que les entreprises aient ou non testé leurs modèles en interne
* Selon le rapport, la Chine réglemente les applications d'IA de manière plus stricte que les modèles de pointe
par Eduardo Baptista
Les principaux développeurs chinois d’IA n’ont rendu publics les résultats des tests de sécurité spécifiques à leurs modèles que pour une infime partie de leurs lancements, selon un rapport du cabinet d’études SemiAnalysis, alors que les inquiétudes concernant les risques posés par les systèmes d’IA avancés ne cessent de croître à l’échelle mondiale.
SemiAnalysis, un cabinet d’études technologiques basé en Californie, a examiné 857 modèles lancés entre 2021 et le 15 septembre par neuf grandes entreprises chinoises spécialisées dans l’IA: Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax et StepFun.
Il a constaté que 31 lancements, soit 3,6 %, étaient accompagnés d’un résultat d’évaluation de sécurité publié pouvant être associé à un modèle spécifique. Seuls neuf, soit 1,1 %, disposaient de tels résultats au moment du lancement ou avant celui-ci, précise le rapport. Les chercheurs n’ont trouvé aucune information relative à la sécurité pour 813 lancements, bien que les entreprises aient pu mener des tests en interne.
SemiAnalysis a précisé qu’elle définissait les informations divulguées comme des résultats spécifiques liés à un modèle nommé — notamment des tests portant sur les sorties nuisibles, la résistance au « jailbreak », la toxicité, la confidentialité, les comportements de refus ou les capacités dangereuses — et ne tenait pas compte des affirmations générales selon lesquelles un modèle avait été entraîné ou évalué en matière de sécurité.
Ces conclusions interviennent alors que les incidents de sécurité impliquant des agents IA autonomes — des systèmes qui effectuent des tâches en plusieurs étapes avec une intervention humaine limitée — ont intensifié le débat mondial sur la nécessité pour les entreprises de ralentir le rythme de développement afin de créer des modèles plus sûrs.
La grande majorité des modèles d’IA capables d’alimenter des agents pouvant mener de manière autonome des cyberattaques sont développés soit par des développeurs américains, soit par des développeurs chinois.
L’Australie a déclaré le mois dernier qu’un agent OpenAI avait piraté un portail gouvernemental dédié à la santé.
Reuters a rapporté la semaine dernière que des agents d’IA chinois avaient démontré leur capacité à tromper les utilisateurs, à contourner les restrictions et à dissimuler des défaillances lors de tests, faisant écho aux inquiétudes soulevées concernant les systèmes américains de pointe.
Le dernier cadre chinois de gouvernance de la sécurité de l’IA identifie des risques, notamment le fait que des modèles obtiennent des autorisations système ou des ressources externes sans autorisation, trompent les évaluateurs, dissimulent leurs capacités et contournent les contrôles de sécurité. Toutefois, selon SemiAnalysis, il n’impose pas d’obligations liées aux capacités des modèles.
Le rapport indique que les règles contraignantes de Pékin régissent principalement les applications et leurs effets sur les utilisateurs, plutôt que d’exiger des développeurs de pointe qu’ils mènent ou publient des évaluations des risques basées sur les capacités d’un modèle.
Le cabinet d’études américain ajoute qu’aucun développeur chinois majeur n’a publié de modèle textuel de pointe accompagné de tests de capacités dangereuses rendus publics, couvrant les risques cybernétiques, biologiques et de perte de contrôle.
Le rapport ne fournit pas de chiffres comparables pour les développeurs américains d’IA. Des entreprises américaines de premier plan, notamment OpenAI, Anthropic et Google DeepMind, ont publié des rapports de sécurité, des fiches système ou des fiches de modèle pour certains lancements majeurs de modèles de pointe.

0 commentaire
Vous devez être membre pour ajouter un commentaire.
Vous êtes déjà membre ? Connectez-vous
Pas encore membre ? Devenez membre gratuitement
Signaler le commentaire
Fermer